메뉴

#긴 문맥 처리

MP
MarkTechPost 41일 전
IMP 8

KV 캐시 압축 기술 경쟁: TurboQuant vs OSCAR vs EpiCache

최근 긴 문맥(Long Context)을 처리하는 AI 모델에서 모델 가중치보다 KV 캐시가 차지하는 메모리 비중이 훨씬 커지는 병목 현상이 발생하고 있습니다. 본 글은 이러한 메모리 문제를 해결하기 위해 등장한 TurboQuant, OSCAR, EpiCache 세 가지 기술의 접근 방식을 분석하며, 이들이 서로 경쟁하기보다는 각자 다른 측면을 보완해 주는 관계라고 설명합니다.

KV 캐시 메모리 최적화 대규모 언어 모델
MP
MarkTechPost 57일 전
IMP 7

미니맥스, 100만 토큰 컨텍스트 지원하는 '미니맥스 M3' 공개

미니맥스(MiniMax)가 최신 AI 모델인 '미니맥스 M3'를 발표했습니다. 이 모델은 미니맥스 스파스 어텐션(MiniMax Sparse Attention, MSA) 아키텍처를 채택하여 최대 100만 토큰의 긴 문맥을 처리할 수 있습니다. 특히 이미지와 비디오 등의 원시 멀티모달리티(Native Multimodality)를 기본 지원하며, 에이전틱 코딩(Agentic Coding)과 컴퓨터 사용(Computer Use) 기능까지 통합된 것이 핵심 강점입니다.

미니맥스 에이전틱 코딩 멀티모달